阿里巴巴宣佈推出千問系列模型 Qwen 3.8-Max。該模型擁有 2.4 萬億參數,並支援多達 100 萬 Token 的上下文窗口。在第三方榜單中,Qwen 3.8-Max 於 Text Arena 排名第 5,在 Vision Arena 排名第 2,測試結果顯示其具備處理編程、辦公、科學研究及長週期任務的運作能力。作為多模態基座模型,它全面支援視覺智能。目前全球開發者可透過阿里雲國際百煉平台的 API 調用該模型,用戶亦能在 AI 辦公智能代理平台 Qwen Work 上測試其功能,而模型權重預計將於短期內對外公佈。
在底層技術方面,Qwen 3.8-Max 基於 Qwen 3.5 開發,採用稀疏混合專家 MoE 架構,並結合混合注意力機制。這項設計旨在平衡模型規模與推理效率,雖然總參數達 2.4 萬億,模型在實際推理時啟動約 950 億參數。官方資料顯示,此架構使模型在處理複雜任務時,相較於同等規模的密集模型能降低計算成本與延遲。在自主編程與長週期執行上,模型在 Frontend Code Arena 排名第 4,具備長時間獨立運行能力。在內部測試中,該模型完成了一個為期 16 天的軟件工程項目開發,建立一個整合用戶反饋與自測數據的自進化 AI 代理框架,產出名為 oh-my-cli 的框架並已開源於 GitHub。
Qwen 3.8-Max 亦被應用於其他專業領域。開發團隊指出,它能復現已發表的研究實驗及設計新方法,並在多模態對話意圖識別挑戰賽中完成分析客服對話紀錄的要求。模型設計涵蓋應用設計、法律文件審查、體育數據分析與建築 3D 建模等工作情境,支援系統級規劃與端到端閉環學習。在多模態智能方面,模型能將文件、電視劇集或長達 100 小時的直播內容轉化為可搜尋的知識庫。團隊透過長週期應用重構基準測試 RecreationBench 進行驗證,結果顯示在黑箱及無法查看原始代碼的情況下,模型能依靠互動式評估與視覺反饋重構應用程式,反映其混合型智能代理的運作特徵。
